第 11 章 · 第三步:指挥 AI 干活

第11章 发起任务后,系统做了什么

从你点下「新建任务」那一刻,到收到成品,中间到底发生了什么。这一章给你一条完整的链路,让你能预判「接下来会看到什么、要等多久、什么时候轮到我」。

阅读约 18 分钟 新手友好 重点:执行时序 / 引擎选择 / 验收

你将学会

先给一句总答案

你点的不是「调用某个人」,而是把活放进一张排班表。系统会按运行模式(要不要自动跑循环)、任务类型、引擎选择(怎么干)、角色配置(谁来干)自动决定后续的一切。你不必指定谁来干,但你可以随时插手改。

你新建任务
→
平台界面写入任务
→
自动运营循环按时间片排班
→
引擎执行loop 或 agent
→
独立验收对照任务描述判定
→
通知你或等你介入

这张图是本章的地图。下面我们按顺序把每一步拆开讲:点击之前系统已决定的事、任务怎么入队、调度器怎么排班、谁来干、一轮里发生了什么、验收怎么判、你什么时候会被叫到、全局怎么重排。最后一节用一个小案例把所有概念串起来。

一、第 0 步:一次点击之前,系统已经决定的事

很多人以为「点了新建任务,AI 就开始干了」。其实在你点击之前,有一整套环境已经配置好了,任务只是落进这套环境里。同一句任务描述,在不同环境里的命运可能完全不同:有的 3 分钟就跑起来,有的一直躺着不动。所以先认识这五件事。

1. 项目运行模式:决定有没有「自动循环」

这是最上面的开关。项目有三个模式,在自动运营控制台「调整运行模式」里是这套叫法:

全自动

AI 自动拆解任务、调度轮次、评审验收,全程自动执行,仅在关键节点通知你。

循环会跑

半自动 默认

AI 自动执行,但在关键决策节点(目标变更、大额支出、对外动作等)由人工确认后继续。

循环会跑

人工审核

AI 产出方案后必须人工审核通过才执行,节奏较慢但最可控。

循环不跑

这是新手最常踩的一个坑

只有全自动 / 半自动会启动「自动运营循环」。选了人工审核(在新建项目向导里叫「手动」),系统不会自动跑循环,你建的任务会一直停在「待执行」——直到你自己去触发它。如果你建完任务发现它纹丝不动,先回来看看这个模式。

2. 执行策略是否已确认

建项阶段,AI 会生成一份「项目执行策略」(目标拆解、关键路径、所需岗位、预算建议、里程碑),需要你确认。这是启动自动运营的一道门槛。官方告警原文是:

告警原文

「未确认策略时,启动自动运营会被拦(/autoops/start 要求已确认策略)。」

换句话说:策略没确认,你连「启动」都点不动。去「引导建项」页面的「项目执行策略」卡里点「确认策略」「完成建项」。

3. 钱够不够:项目预算与 AI 运行预算

任务是要花钱的(模型按 token 计费)。系统在每一轮开始前都会先看一眼预算余额:

预算水位系统会做什么你该做什么
正常照常跑什么都不用做
达 80%发「预算预警」通知,进入降级运行评估要不要补预算
超限熔断:暂停循环,等补充预算去自动运营控制台点「恢复」或「启动」

补充一点:预算熔断是「项目 AI 运行预算」这一层;它和平台真实账本的余额熔断是两本账,别混淆。计费明细页的「已熔断 / 预警」标签就是这一层的状态。

4. 已经有哪些智能体、它们会什么

任务最终要落到某个角色(岗位)头上执行。这个角色决定了用哪套提示词、带哪些技能白名单。如果项目里还没建 Agent,系统会用默认角色兜底,但效果不如你配好的专业角色。所以:想让活儿干得专业,先建好对应的 Agent。

5. 哪些功能开关开着

设置页「功能管理」里有一排开关,界面按中文名展示、并分为「基础 / 高级」两组:自动构建部署(deploy)、通知中心(notification)、自动备份(backup)、自动报告(report)、智能报告(auto_report)、项目模板(project_template)、营销自动化(marketing)、营销自动化引擎(marketing_engine)、社交媒体管理(social_media)、战略规划(strategy)、渐进式信任(trust_model)、冲突仲裁(arbitrator)、资源治理(resource_governor)等。开关关着的功能,相关任务即使建了也不会真的产生对外动作。

两点容易看错:其一,「自动报告」(report)和「智能报告」(auto_report)是两个不同的开关,别把它们当成同一个;其二,「渐进式信任」「资源治理」属于安全底线项,界面上置灰、不可关闭,后端也会拒绝关闭请求,这是刻意的保护而非故障。系统遇到未登记的新开关 key 时会归入「其它」,不会凭空隐藏。

别小看这一排开关,它们决定「AI 有没有真正对外出手的权限」:比如 marketing 关着,AI 就算写出了营销文案,也不会真的去发布;deploy 关着,AI 不会自动把代码构建部署上线。所以如果你发现「文案写了却没发出去」「代码改完了却没上线」,先来查这里——很可能不是任务失败,而是对应开关没开。

新手建议:先只开确实需要的(比如通知、报告),等流程跑顺了再逐个打开「对外动作」类的开关,避免 AI 在你还没准备好时就替你做决定。

一句话记住这一节

任务不是凭空执行的,它落在一套已配置好的环境里。模式、策略、预算、Agent、开关,这五样都在你点击之前就位。任务卡住时,先回头查这五样。

二、第 1 步:任务入队(你点下「新建任务」之后)

自动运营 › 任务管理 › 新建任务

点开「新建任务」,弹窗里的字段不多,但每一个都会影响任务后面的命运。完整列一遍:

字段填什么影响
任务名称 必填如「市场定向调研」列表展示、验收报告引用
描述一句话说清要什么、什么算做完验收的唯一依据(见第六节,界面没有单独的验收标准输入框)
任务类型通用任务 general / 新建软件工程 eng / 软件修改 modeng、mod 会走软件工程向导,工作区按项目维度共享
优先级P0 - 紧急 / P1 - 高 / P2 - 常规 / P3 - 低排班顺序参考,P0 排前面
时间片权重1–10 的整数每轮能分到多少时间(下面第三节细讲)
引擎类型循环执行 loop / Agent 智能体 agent(界面选项显示为「Agent 智能体(Agent 引擎)」)用哪种方式干(第四节细讲)
AI 模型placeholder「路由自动」留空即按路由自动选模型;也可指定
关联软件工程mod 类型必填软件修改挂到哪个源工程上
时限(秒)默认 7200单轮执行上限,超时强杀后进入下一轮
角色 IDplaceholder「指派 Agent 角色 ID(可选)」由哪个岗位的提示词与技能来干
提示词模板placeholder「任务执行提示词模板」任务级提示词,覆盖角色级、项目级

填完点「确定」,立刻会发生三件事:表单校验通过 → 任务写入 → 任务出现在列表里,状态是 待执行 pending。

然后,就暂时停下了。任务不会瞬间开跑,它在等调度器在下一轮把它选中。

「不发生的什么」比「发生的什么」更重要

点完按钮之后不会发生:不会立刻弹出一个 AI 开始跟你对话,不会立刻产生日志,不会立刻花钱。真正开跑的时点是「调度器选中它」,通常要等到下一个轮次。如果你建完任务就去日志面板刷新,多半什么都看不到——这是正常的。

为什么会一直「待执行」

状态长期停在 pending,几乎都是下面几种原因,按出现频率排:

  1. 项目没启动

    项目状态不是「运行中」。去项目详情页点「启动」。

  2. 自动运营没开

    项目在跑,但没启动自动运营循环。去自动运营控制台点「启动」。

  3. 运行模式是人工审核

    这个模式不启用循环,任务必须你手动触发。

  4. 任务在排队

    循环在跑,但这一轮排到别的任务,你的任务还没轮到。看运行轮次页确认。

  5. 任务自身被暂停

    任务的 status 被置成了 paused,去列表点「恢复」。

这五种原因的详细排查步骤,见附录 B 的排查树。

软件工程类任务多一个前置阶段

任务类型选「新建软件工程」或「软件修改」时,建完之后不会立刻进入排班,而是先走一段规划阶段:系统先把它拆成可执行的工程步骤(动哪些文件、分几步、怎么验证),方案定了再交出去干。所以这类任务刚建完的状态可能是「规划中」,而不是「待执行」——这是正常的。

两个常见疑问,一次说清:

还要记住一点:软件工程类任务的设计文档是按软件名称分目录隔离的——每个「新建软件工程」任务的设计文档写进自己软件名对应的子目录({项目工作区}/{软件名称}/),各写各的 PRD/TAD,不会互相覆盖。软件修改任务读写的也是它「关联软件工程」对应的那个文档目录。注意区分:隔离的是文档;代码工作目录仍是项目级共享的(整个项目一个代码库),所以同一个项目里做两个互不相干的软件时,代码文件仍可能互相看见、互相影响——真要完全隔离,建议拆成两个项目。这类任务更适合用循环执行引擎——它必须能真正读写工作区里的文件。

三、第 2 步:调度器排班——时间片是怎么回事

这是整套机制里最「反直觉」、也最值得花五分钟搞懂的部分。搞懂它,你就能预判「我的任务大概多久轮一次」。

3.1 排班表长什么样

系统维护一张排班表,默认有 10 个时间片(你可以理解成 10 个工位)。每个时间片里放一个任务编号(或者空着)。任务通过「时间片权重」占据多个时间片:权重填 5,就占 5 个工位。

假设你有三个任务:

任务优先级时间片权重占用的工位
t1 上线支付回调P0 - 紧急50、1、2、3、4
t2 写营销邮件P1 - 高35、6、7
t3 整理周报P2 - 常规28、9

每推进一轮,系统从下一个时间片开始,往后找到第一个「还没完成」的任务,把它交出去执行。起始位置每轮往后挪一格,任务就自然轮流获得处理时间。

3.2 三个任务 × 10 轮的排班示意

假设三个任务都没完成、没有新任务插入,10 轮的实际选中情况是这样的:

轮次起始时间片选中任务这一轮谁在干活
第 1 轮0t1上线支付回调
第 2 轮1t1上线支付回调
第 3 轮2t1上线支付回调
第 4 轮3t1上线支付回调
第 5 轮4t1上线支付回调
第 6 轮5t2写营销邮件
第 7 轮6t2写营销邮件
第 8 轮7t2写营销邮件
第 9 轮8t3整理周报
第 10 轮9t3整理周报

10 轮下来,t1 拿到 5 次、t2 拿到 3 次、t3 拿到 2 次——正好等于它们的时间片权重。这就是「时间片权重」的准确含义:它不是你想象的「分多少秒」,而是「每 10 轮里占几轮」。

为什么用时间片,而不是排队做完一个再做下一个

因为真实项目里,任务往往是并行推进、需要往复迭代的(写完要等反馈、改完要重跑)。如果一次只做一件、做完才做下一件,一个卡住的长任务会拖垮全局。时间片让每个任务都能周期性获得关注:谁更急,就给它更多片。设计原文见 TAD-v2/04(附录 D 有摘录)。

3.3 任务完成后会发生什么

任务一旦被标记完成,它的时间片会被自动跳过。上例里如果 t1 在第 5 轮后完成了,那么第 6 轮起,起始片 5、6、7 仍指向 t2,而原本落到 t1 的空档会由后面的任务补上——你的其他任务会「提速」。这也是为什么先干完一个任务,往往能让剩下的任务跑得更快。

3.4 「为什么我建了任务但它在排队」以及「怎么更快」

排队是正常现象。你想让它更快被处理,有四个办法,按推荐度排:

✅ 这样做

  • 提高时间片权重:从 1 提到 3–10,它在每 10 轮里占的轮数变多。
  • 提高优先级:P2 改 P1 或 P0,排班时被排在前面。
  • 减少同时进行的任务数:任务少,每个分到的轮数自然变多。
  • 缩短单轮时限:长任务把单轮卡满,减小「时限(秒)」能让轮转更快。

❌ 别这样做

  • 不要把所有任务都调成 P0 权重 10——等于没调,反而整体变慢。
  • 不要为了「让它快点」而反复暂停/恢复,这不会插队。
  • 不要在预算已预警时猛加任务,熔断后全部停摆。

四、第 3 步:谁来干——引擎与角色的两级决定

「我发起任务,是自动调用智能体还是怎样?」——答案分两层:引擎决定「用什么方式干」,角色决定「由哪个岗位的提示词与技能来干」。这是两个独立的决定,很多人都混成了一件。

4.1 引擎决定「怎么干」

系统有两套干活的引擎,人话解释是:

循环执行 loop 默认

派一个外部执行工具去跑(类似一个能干活的命令行助手),适合复杂、编码、构建、长时任务。

它能在你的项目工作目录里真正读写文件、跑命令、改代码,产出完整交付物。

Agent 智能体 agent

系统内部直接调 AI + 工具调用,不开外部进程,适合信息整合、接口调用、快速任务。

反应快、成本低,但不擅长交付完整软件。

系统怎么选?有一条明确的优先级:

任务级任务里指定了引擎
→
角色级角色 RunConfig 里配的引擎
→
项目默认
→
兜底 loop

也就是说:任务里明确指定了就用它;没指定就看执行角色有没有配;还没有就用项目默认;全都没有,兜底用循环执行。

4.2 你没指定时,系统怎么猜

任务没写引擎类型时,系统会按描述里的关键词做一次启发式预测:

界面上的官方警告,务必读一遍

在新建任务弹窗里,当任务类型是「新建软件工程 / 软件修改」、且引擎类型选中「Agent 智能体」时,界面会弹出一条警告(原文):

「Agent 引擎可能无法完成软件交付,仅适合简单项目,建议使用循环执行」

翻译成决策建议:要交付软件、要产出可运行的东西,就用循环执行(loop);只是问一句、汇总一份、发个通知,用 Agent 智能体(agent)。不确定就用 loop,它是安全的默认值。

4.3 角色决定「谁来干」

引擎定了「方式」,角色定了「人」。角色的作用有两块:

打个比方:引擎是「派去的是外包工人还是内部员工」,角色是「派了个会计还是派了个程序员」。同样是「内部员工」,会计不会去改代码。

4.4 两级决定对照表:10 个典型任务会落到哪

你的任务会落到哪个引擎由谁干(角色)
新建软件工程:实现 JWT 登录模块loop(编码/长时)全栈开发角色
修改现有代码里的一个 Bugloop(软件修改 mod)全栈开发角色
把本周销售数据汇总成一份报告agent(信息整合)数据分析角色
翻译一份英文产品说明成中文agent(快速任务)内容角色
给 20 个客户批量发跟进邮件agent(工具调用为主)销售/营销角色(需人工审核外发)
长时构建并部署上线到服务器loop(构建/部署)运维/开发角色
基于知识库回答「我们的目标客户是谁」agent(问答/检索)通用业务角色
生成 3 篇英文营销邮件文案agent(生成文案)营销内容角色
跑单元测试并修复失败用例loop(测试/编码)全栈开发角色
竞品调研并整合成一份对比表agent(搜索/整合)市场研究角色
描述很含糊,不知道算哪类loop(兜底)按角色 ID,未指定则默认角色
想省钱的读者看这里

agent 引擎不开外部进程,通常更便宜更快;loop 引擎干得重、花得多。如果你的任务其实是「问一句、汇总一下」,把它建成 agent 往往能省下不少 token。反之,你拿 agent 去交付软件,多半会得到一堆「看起来像但不完整」的产出。这个取舍见附录 C。

4.5 想换引擎,或一开始就定死,怎么做

你有两个时机可以定引擎,而且都可以事后改:

一个实用建议:拿不准的任务先别指定引擎,让系统的关键词启发式自己判断;等你发现它总选错,再手动定死。这样既省心,又能在需要时精确控制。反过来,如果是「一定要交付软件」的任务,建议一开始就明确指定循环执行,省得它被猜成 agent 白烧几轮。

五、第 4 步:一轮里到底发生了什么(最重要的一节)

现在进入正题:调度器选中你的任务,接下来这一轮(一班)里,系统按顺序做这几件事。请对照着看,每一小步我都标注了「你在哪个页面能看到」。

① 组装提示词任务+接力+角色+知识库
→
② 调用引擎执行产生日志
→
③ 消耗 token 记账
→
④ 生成交接班记录
→
⑤ 完成判定
→
⑥ 撞上人工节点就等你

5.1 组装提示词

在把活交出去之前,系统会先「把这一轮要说的话拼好」。拼进去的有五块:

拼进去的内容它是什么为什么需要
任务描述你在任务里填的 name / desc告诉它这一轮干什么
接力摘要上一轮留下的「本轮目标 / 已完成 / 未完成点 / 下一步」让它接得上,不用每次从零理解
角色设定这个岗位的提示词(按任务级 > 角色级 > 项目级继承)决定它用什么身份、什么风格干
知识库检索结果从项目/公司知识库里按相关性取出的资料让它基于你的资料回答,少瞎编
优秀案例历史上被采纳的优质产出(动态 Few-Shot)给它看范例,产出更贴近你的口味

这一步你在界面上看不到直接的东西——它是后台组装。但你会在日志里看到它的「痕迹」:如果提示词里带了知识库内容,AI 的回答通常会引用到你的资料。

5.2 调用引擎执行,期间产生日志

引擎开始干活。你在这个阶段应该去的地方是:

自动运营 › 运行轮次 › 选中某一轮 › 日志

日志面板里每一条都带一个标签,标签是英文的,这里逐个给你翻译:

日志标签人话解释
assistantAI 的正式输出(你会读到的「正文」)
thinkingAI 的思考过程(它怎么想的,可能比较啰嗦)
tool_useAI 决定调用某个工具(比如读文件、跑命令、发请求)
tool_result那个工具返回的结果(成功或报错)
user投喂给 AI 的输入(多半是系统组装的那段提示词)
system系统级信息(环境、配置、警告等)
summary本轮的收尾摘要(也就是下一节要讲的「交接班记录」)

标签看着多,读日志的顺序其实很简单,按这四步看就够:

  1. 先看 user,确认「这轮让它干什么」

    这一段是系统拼好的提示词。如果这里就已经跑题(比如漏带了关键资料、角色选错了),后面它再努力也白搭——问题出在配置,不在 AI。

  2. 再看 tool_use / tool_result,看它「查了什么、拿到什么」

    工具调用失败、权限不够、文件找不到,这类报错通常就出现在 tool_result 里。排错第一现场在这里。

  3. 然后看 assistant,看它「交出来什么」

    这是你真正会读到的正文,也是验收 Agent 主要看的部分。判断任务有没有跑偏,主要看这一块。

  4. 最后看 summary 和 system,看它「自评干到哪 + 花了多少」

    summary 是它给自己写的交接班记录;system 里有本轮用了多少 token、跑了多久。

日志是实时推的

运行轮次页和日志面板会通过 WebSocket 实时推送日志,你不用手动刷新。如果连接不稳,页面会在 3 秒内自动回退到定时轮询,你看不到「断流」,只会看到刷新稍慢一点。面板上还会有一行小字告诉你当前是「自动刷新中,内容会随轮次更新」还是「已暂停自动刷新,内容可能已过期」——看到后者时,先手动刷新再读,别拿旧内容下判断。

「暂无日志」和「加载失败」是两回事

面板把两种情况分开显示,别混淆:「该轮次暂无日志(任务开始执行后自动生成)」是正常空态——这一轮还没产生日志(底层接口返回 404,按空态处理),等它跑起来就有;「日志加载失败(HTTP 状态码),请稍后重试;若持续失败请检查实例是否在线」才是真出错,说明请求拿到了非 404 的错误状态,这时先确认项目实例是否在线,再重试。

5.3 消耗 token,自动记账

这一轮 AI 说了多少字、读了多少字,都折算成 token,按单价计费:

输入单价
¥1
每百万 token · 你喂给 AI 的内容
输出单价
¥2
每百万 token · AI 产出的内容
缓存读取单价
¥0.02
每百万 token · 复用的上下文,极便宜
记账位置
2 处
计费明细 + 项目账本

单价不是死的,可以在项目详情页「运行配置 → 定价(元/百万 token)」里改。花出去的钱会写进两个地方:一是「计费明细」页(累计花费、输入/输出 Token、预算已用),二是项目账本(虚拟核算)。

计费明细里有一个「估算」的口径,别当发票

计费明细页有一条 tooltip 原文:「其中包含按文本长度估算的兜底计费(上游未回 usage 时产生),非精确账单,请勿直接作为账单核销」。意思是:极少数情况下上游没返回精确用量,系统会按文本长度估算一笔。看趋势可以,别拿它对账。

5.4 执行结束,生成本轮的「交接班记录」

一轮干完,系统不会让这轮的成果随风而去。它会把「本轮目标 / 已完成动作 / 未完成原因 / 下一步建议」存成一份交接班记录。下一轮轮到同一个任务时,这份记录会被自动拼进提示词——这就是 5.1 里说的「接力摘要」。

设计上有一条硬约束:如果这一轮没干完,交接班记录必须保留「未完成点 + 下一步」,保证下一轮能续上,而不是每次重新开始。

为什么要接力,而不是一轮干到底

因为一个复杂任务(比如写一个模块)可能要几十轮、跨越好几个小时甚至几天。中间可能被人工审批、预算暂停、实例重启打断。接力摘要让 AI「睡一觉回来还记得干到哪」——这是长期运行的命脉。设计理由见附录 D。

5.5 判断是否完成

怎么算这一轮把任务干完了?规则很朴素:系统看这一轮输出的末尾有没有出现完成标记。出现了,就进入验收;没出现,就说明还没干完,下一轮接着干(带着交接班记录)。

进阶:这个「标记」具体是看哪里

系统会在本轮输出的末尾一小段(约 50 字以内)里找约定的完成标记。之所以只看末尾,是为了避免正文里讨论到「完成」两个字就被误判为干完了。

这个细节对你的意义:如果你自己写提示词模板,别让任务的收尾语把标记的位置挤掉(比如在标记后面又加一大段总结)。想让它干净收尾,提示词里明确要求「最后单独一行输出完成标记」最稳妥。

这条规则对你有直接影响

因为「完成」是靠一个约定好的标记来判定的,所以:不要指望 AI「差不多写完了」就算完成。它是按标记来的。这也解释了很多人看到的「任务跑了很久还在跑」——不是卡住了,是还没到收尾那一刻。你可以在日志里找 summary 标签,看看它每轮觉得自己干到哪了。

5.6 撞上人工节点 / 预算预警 / 敏感动作,就停下来等你

一轮的执行不是一路畅通的。有三种情况会让它主动停下来等你:

人工处理节点

AI 要你确认某件事(审核文案、批准外发等),就建一个节点等你。

去「人工处理节点」页看。

预算预警 / 熔断

预算到 80% 发预警;超限直接熔断暂停。

去「计费明细」和「自动运营控制台」看。

敏感动作

对外发布、删除、付费、打款等被拦下,转人工。

去「人工处理节点」页看。

注意一个细节:你点了「暂停」之后,系统不会杀掉正在执行的那一轮,而是等它跑完再停。这是故意的——半路掐断会丢上下文。恢复后从下一轮继续,进度不丢。

5.7 中断之后还能接上吗——续跑机制

长期项目难免遇到中断:实例重启、你手动暂停、预算熔断。很多人的担心是「停了这么久,是不是要从头再来」。答案是不用,但系统会按停机时长分档处理:

中断时长系统怎么处理你看到什么
很短(约两天内)直接干净续跑,不额外检查恢复后接着上一轮往下走,几乎无感
较长(数天到一个月)先做一次「环境漂移检查」:比对代码有没有被改、依赖装没装、接口凭证是否还有效、数据结构变没变、知识库更新没有恢复时可能多出一份检查结论
很久(超过一个月)认为原计划可能已过时,重新规划任务集,而不是硬续会看到任务被重排或新增

为什么要做「环境漂移检查」?因为 AI 上一轮是在某个环境里干到一半的。如果中间有人改过代码、换过凭证、动过数据结构,它拿着旧记忆接着干就会出错。先检查一遍再续,是防止「带病续跑」。这也是为什么长期停摆后恢复,前几轮可能看起来在「重新摸底」——那是正常的安全动作,不是它在摸鱼。

进阶:续跑时系统到底比对了哪几项

环境漂移检查会逐项比对:代码仓库有没有新提交、运行依赖是否与上一轮一致、对外接口凭证是否仍然有效、数据结构版本有没有变化、知识库有没有新增资料。任何一项漂移达到阈值,就会从「直接续跑」降级为「带调整续跑」;漂移过大则干脆重新规划。

对普通读者来说,你只需要记住:恢复后如果任务被重排,通常是系统判断环境变了,而不是你哪里设置错了。

六、第 5 步:验收——为什么不是干活的 AI 自己说了算

任务跑到完成标记之后,不会直接算完成。它会先过一道验收,而且这道验收是由一个独立的验收 Agent做的——这就是常说的三权分立:干活的人、验收的人、批准的人,三方分开,防止「自己给自己判及格」。

角色谁在担干什么
执行(R)员工 Agent(任务指定的角色)真正干活、产出
验收独立验收 Agent(与执行者不同的角色)对照任务描述判定合格与否
批准(A)负责人 / 管理者 Agent 或你本人高风险产出必须人工批准

6.1 三种验收结论,各触发什么

通过 pass 完成

任务标记完成,记录总轮次/总耗时,发「任务完成」通知,后续时间片跳过它。

返工 redo 重做

任务重新回到调度队列(不标记完成),验收意见注入下一轮提示词,反复重做超过上限会升级人工。

驳回 reject 升级

任务转失败,升级到管理者 Agent 或人工处理节点,由人来判后路。

6.2 去验收记录页看「两个 ID」

自动运营 › 验收记录 › 详情

打开一条验收记录的详情,你会看到两个关键的 ID:

列表上你还看得到「结论」(通过 / 返工 / 驳回)、「评分」「抽样」「成本」「人工状态」(待审批 / 已批准 / 已拒绝)。评分和报告就是验收 Agent 给出的依据。

另外有个「抽样」标签:低风险任务不会每次都验收,可能会按比例抽样(抽不中的本次直接放行,零成本);高风险、对外发布、财务、合规类任务则强制全量验收,必要时还要人工批准。验收强度按任务风险分级,大致是这样:

任务风险验收强度要不要人工批准
关键 critical全量验收必须人工批准
高 high全量验收视情况(对外动作、财务类需要)
中 medium全量验收一般不需要
低 low按比例抽样(约三成)不需要

这就解释了为什么有些任务「跑完就完了」,有些却会停下来等你批——差别在风险等级。所以重要任务不要含糊描述,写得越像「关键任务」,系统给它的把关就越严。

最重要的一句提醒:什么算「做完」必须写进描述

当前界面上没有一个单独让你填「验收标准」的输入框(该字段在接口层存在,但没开放到界面)。验收 Agent 判定时,主要依据是你写的任务描述。而且任务描述创建之后不能修改——所以更要一次写准:「什么算做完」务必写进任务描述里,而且要可验证。

反面例子:「优化一下官网」——验收 Agent 无法判定合格与否。
正面例子:「产出 3 篇英文营销邮件,每篇 200 词以内,包含明确 CTA 链接,保存在项目 marketing 目录下」——可逐条对照。

七、第 6 步:通知与你的介入点

前面说过,系统会在关键处停下来等你。但「等你」之前,它得先通知到你。

7.1 你会收到什么

通知中心里,通知按类型分(原文标签):

类型含义通常什么时候出现
budget_alert 预算预警钱快不够了预算达 80% / 熔断时
approval_required 审批请求有件事等你点头撞上人工节点 / 敏感动作时
task_complete 任务完成某个任务验收通过了验收 pass 后
milestone 里程碑阶段成果达成目标树 KR 达成时
campaign_update 营销更新营销活动有进展开营销自动化时
system 系统通知系统级消息异常、暂停、终止等

通知的渠道有:站内通知中心、飞书、Telegram,以及移动端审批页(手机上直接「批准 / 拒绝」)。优先级分 urgent 紧急 / important 重要 / normal 普通 / info 信息,紧急的会走多渠道推送。

7.2 你的四种介入动作

当系统等你时,你手上的牌其实只有四张。逐个说清「什么时候用哪张」:

  1. 审批(批准 / 拒绝)

    什么时候用:收到「审批请求」,AI 停在人工节点上。
    去哪做:人工处理节点页点「确认完成」;或打开「移动审批」页(手机端点「批准 / 拒绝」,可填审批意见)。
    效果:批准 → 任务继续推进;拒绝 → 该动作终止,转人工决策后续。
    点了没反应?不会。如果任务/节点已经不在待审批状态(状态已变更、已被他人处理、或对象不存在),系统会返回明确的中文错误(例如「任务当前状态不可审批(仅 waiting_approval 可审批;任务不存在或状态已变更)」),而不是显示成功却没改动任何东西。

  2. 注入信息(纠偏)

    什么时候用:AI 理解偏了,或你有新要求,但不想推翻任务重来。
    去哪做:到「智能体中心 → 任务」对运行中的任务点「注入」,输入新信息(placeholder「运行中注入的新信息」);也可以把补充要求写进任务的「提示词模板」(自动运营的任务列表点「编辑」可改)。
    效果:新信息会在下一轮拼进提示词,AI 下一轮就按新信息调整。
    要特别注意:任务的描述在创建之后不能改——「编辑」只开放优先级、引擎、时限、模型、提示词模板这几项。所以「什么算做完」这类关键信息,建任务时就得一次写准。

  3. 暂停 / 恢复

    什么时候用:你想先停一停看清楚,或者不想再烧钱。
    去哪做:项目详情页「暂停 / 恢复」;自动运营控制台「暂停 / 恢复」;任务列表里对运行中的任务点「暂停」,对已暂停的点「恢复」。
    效果:当前轮跑完再停(不杀在途进程);恢复后从下一轮继续,进度不丢。

  4. 调整预算

    什么时候用:收到预算预警或熔断,且你决定继续投钱。
    去哪做:项目详情页「预算明细 → 调整预算」;或在自动运营控制台改 AI 运行预算。
    效果:补足预算后点「恢复」,循环继续。注意兜底暂停是持久状态(跨重启保留),必须人工处理后手动恢复;此时页面上指向的是「恢复」而不是「启动」。

7.3 SLA 与超时升级

人工节点不是无限期等你的。每个节点有 SLA(超时秒数)和处理人。如果你没在 SLA 内处理:

节点的「通道」分三种:红(强制人工,如对外发布、打款)/ 黄(敏感,需确认)/ 绿(例行,通知即可)。「自主级别」分 L0–L3:L0 全自主、L1 通知不等、L2 一键确认(默认)、L3 强制审核。级别越高,AI 越自由;级别越低,越依赖你。

7.4 通知会不会太多?

不会。系统按优先级做分渠道路由:紧急(urgent)级别的通知会多渠道同时推送(站内 + 飞书 / Telegram + 移动端),确保找到你;普通级别的则以站内通知中心为主,你有空再翻。原则就是一句话:必须现在拍板的,主动找到你;可以先放放的,安静待在通知中心。

如果你不确定有没有漏掉什么,打开「通知中心」扫一眼就行——它是所有通知的兜底收件箱:哪怕某个外部渠道没送达,站内这条也一定在。按类型过滤,几秒钟就能看完。另外,某个通道暂时没配(比如还没接飞书)时,系统会降级为站内提示,不会让通知凭空消失。

八、第 7 步:轮次推进与全局重排

你已经理解了单轮和验收,现在把它放大到全局。整个项目是一个不断推进的循环,每一轮做上面那一套。除此之外还有两种特殊轮次,是你看到「界面变化」的来源。

8.1 任务轮:按时间片轮流推进

绝大多数轮次是任务轮——就是第 4 步讲的那一套,按排班表轮流选中任务执行。

8.2 review 轮:全局重排,你会看到「任务变了」

每推进一定轮数(默认距上次 review 达 20 轮),或当所有任务都完成时,系统会插入一个 review 轮。这一轮不干活,而是让 AI 停下来审视全局(看代码提交记录、进度、预算、收益),然后重新排布任务集与时间片。

看到「任务顺序变了、多了新任务」,是正常的

很多人被这个吓到:明明没动过任务,怎么列表里多出来几条、顺序也变了?这是 review 轮在起作用——AI 觉得该加新任务、该调顺序、该改权重,就会重排。重排前系统会校验(任务 id 不重复、优先级合法、时间片合法等),校验不过就保留原排班,下一轮重试,不会把排班弄坏。

手动触发 review 的能力:目前后台已经具备,但界面上还没有直接按钮(部分可用)。所以现阶段你主要靠它自动触发。

8.3 free 等待:全干完了,它也不空转烧钱

如果任务全完成了(或者任务集是空的),系统会进入 free 等待模式:不再跑深度任务,只做常规检查,按间隔再 review。这个状态下不消耗 LLM。系统会给你发一条通知,原文是:

空闲等待通知原文

「项目已完成全部任务并空闲等待 N 轮(不再消耗 LLM)。如需继续运营,请注入新信息并触发 review 重排任务」

翻译成人话:活儿干完了,我先歇着,不花钱了。你想让它继续干,就注入新信息(给任务补充要求)或触发一次 review,让它重排任务集。

8.4 我该什么时候做什么:时间轴

你看到的状态意味着什么你现在该做什么
任务待执行 pending,一直不动循环没跑 / 在排队查运行模式、自动运营开关、轮次页
轮次运行中 running正在干活可以看日志,什么都不用做
人工节点「待处理」它在等你尽快去「确认完成」或「批准」(注意 SLA)
预算「预警」标签钱到 80%评估补预算
预算「已熔断」循环已暂停补预算 → 点「恢复」
验收「返工 redo」产出不合格,在重做看验收报告,必要时改任务描述
验收「驳回 reject」升级人工了去人工节点拍板
通知中心「空闲等待」活儿干完了注入新信息或触发 review 继续
出现兜底保护暂停横幅(控制台「项目已因兜底保护暂停」/详情页「自动运营已因兜底保护暂停」)连续失败触发了兜底查日志找原因,处理后点「恢复」

8.5 轮间间隔:为什么不是连轴转

你可能会发现,两轮之间有一段空白期,不是一停就立刻接着下一轮。这是故意的节流。轮与轮之间默认有约 60 秒的间隔,它有三个作用:

所以「下一轮怎么还没开始」通常不是故障,是在等间隔。真正要警惕的是轮次号长时间不推进、又没有任何通知——那才需要回去查附录 B 的排查树。这个间隔可以在项目详情页「运行配置 → 调度配置」里调(对应「默认间隔(秒)」一项)。

8.6 轮次列表为什么只显示最近一段

项目跑久了,轮次会有几百上千条。系统只保留最近一段轮次历史(大约最近 30 轮),更早的会被滚动清理。这不是丢数据,是控制体积的常规做法。

对你的影响是:想回溯早期某一轮到底发生了什么,要趁它还在列表里的时候看。如果你需要长期留档,建议在任务或项目层面定期把产出导出,或把重要结论沉淀进知识库——知识库不会被轮次清理影响。这也解释了很多人的疑惑:「我明明记得跑过上百轮,怎么列表里只剩几十条?」——属正常清理。

九、一次完整案例走查:给独立站写 3 篇英文营销邮件

把前面所有概念串一遍。假设你是一个跨境电商独立站的 OPC 创业者,运行模式是半自动,自动运营已启动,项目预算充足。你新建了这样一个任务:

任务描述示例(可复制改)

为我的【家居收纳类独立站】产出 3 篇英文营销邮件:分别面向「购物车放弃用户」「首单新客」「复购老客」三类人群;每篇不超过 200 词,包含一个明确 CTA 链接占位符,语气友好专业;产出保存到项目文档区,文件名 mail-1/2/3.txt。

下面是「典型情况」下接下来会发生什么(时间是量级示意,实际因模型与项目而异):

  1. 10:00 · 点击「确定」,任务入队

    任务状态变成 待执行 pending,出现在任务管理列表。此刻没有日志、没有花费。你在日志面板刷新看不到东西——正常。

  2. 10:03 · 第 1 轮:调度器选中它

    当前排班轮到它。系统组装提示词(任务描述 + 角色设定 + 从知识库检索到的「产品卖点」资料),交给引擎执行。因为描述里是「生成文案」,系统多会选 agent 引擎。

    你在界面看到:运行轮次页出现一轮,状态 运行中;日志面板开始滚动出 assistant / thinking / tool_use 条目。

  3. 10:14 · 第 1 轮结束,没完成

    输出末尾没有出现完成标记,所以不算完成。系统生成本轮交接班记录:「已完成:邮件 1、2 草稿;未完成:邮件 3 与统一 CTA;下一步:补齐第 3 篇并统一格式」。

    你在界面看到:日志里出现一条 summary 标签,内容就是上面那段。

  4. 10:15 · 轮间短暂间隔后进入下一轮

    如果排班表里还有别的任务,会先轮到别的任务;这里假设只有这一个任务,于是第 2 轮又轮到它。

  5. 10:20 · 第 2 轮撞上人工节点,停下来等你

    AI 认为需要「确认邮件里的 CTA 链接指向」且这属于对外动作,于是创建一个人工处理节点(可能是黄通道,L2 一键确认),任务推进暂停等待。

    你在界面看到:通知中心出现「审批请求」;人工处理节点页出现一条「待处理」,带通道、SLA、处理人;你也可以在手机上打开「移动审批」直接批准。

  6. 10:25 · 你批准

    你点「批准」(或人工节点页点「确认完成」)。节点状态转「已完成」,任务恢复推进。

  7. 10:40 · 第 3 轮:出现完成标记,进入验收

    这一轮输出末尾出现完成标记。系统触发独立验收 Agent(和写文案的不是同一个 Agent)。

    你在界面看到:验收记录页新增一条,结论暂未定,评分与报告随后写入。

  8. 10:42 · 验收返工(本次故意安排一次 redo)

    验收 Agent 对照你的任务描述发现:只产出了 2 篇(描述要求 3 篇),CTA 也没统一。结论 redo 返工,理由写进报告。任务回到调度队列,验收意见注入下一轮提示词。

    你在界面看到:验收记录结论「返工」,报告里逐条列了未达成项。

  9. 11:05 · 第 4 轮:带着反馈补齐

    这一轮提示词里带了上一轮验收的返工理由,AI 补齐第 3 篇并统一了 CTA。再次出现完成标记 → 再次验收。

  10. 11:07 · 验收通过,任务完成

    结论 pass 通过,任务状态转「已完成」,记录总轮次/总耗时,发一条「任务完成」通知给你。

    你在界面看到:任务列表状态「已完成」;验收记录结论「通过」,执行者与验收 Agent 是两个不同 ID;计费明细里能看到这个任务这几轮花掉的钱。

整个链路约 1 小时出头(含一次人工审批等待)。你全程只做了一件事:点了一下「批准」。其余都是系统按排班表自动推进的。

这个案例想教你什么

你会注意到:返工不是失败,是正常质量把关;人工节点不是卡壳,是设计上要你拍板;钱是按轮次一点点花的,不是一次性扣掉。理解了这三点,你就不会一看到 redo 或「待处理」就慌。

十、什么时候「不自动」:人工审核模式下的链路

前面讲的都是全自动 / 半自动下的自动链路。如果你选的是人工审核(新建项目向导里叫「手动」),链路完全不同:

环节全自动 / 半自动人工审核(手动)
自动运营循环启动,自动一轮轮跑不启动
任务怎么开始调度器自动选中靠你手动触发
轮次推进自动按时间片推进你点一次,跑一次
review 重排≥20 轮或全完成时自动触发不自动触发
预算熔断轮前自动检查每次执行时检查
适合谁想让 AI 自己往前推想看清每一步、红线多的团队

一个容易踩的坑:你在控制台把模式从「半自动」改成「人工审核」时,界面会提示:

切换提示原文

「切换后将暂停自动运营循环,仅保留人工审核驱动的执行,可在之后重新启动或调整」

也就是说,切过去之后循环会停。想让它重新自己动起来,得切回全自动 / 半自动再启动。

人工审核模式下,一次任务是这样跑的

因为少了自动调度器,人工审核模式更像「你按一下、它动一下」:

  1. 你建任务

    和平时一样,填描述、优先级、角色,建完状态是「待执行」。

  2. 你手动推动它

    循环不跑,任务不会自己开始。你需要通过任务列表里的操作把任务推向执行,它才会真正开跑。

  3. 跑一轮,产出交给你审

    AI 按当前任务设定执行一轮,产出方案或结果,然后等你审核。

  4. 你审核通过才继续

    审核通过,任务才进入下一步或下一轮;不通过就退回修改,反复直到你满意。

一句话记住差别:全自动 / 半自动是「系统推着你走」,人工审核是「你推着系统走」。红线多、对外动作谨慎、希望每一步都亲眼确认的团队适合后者;想省人力、让 AI 自己迭代的选前者。

模式可以中途改

三种模式不是建项时一锤定音——你可以在自动运营控制台「调整运行模式」里随时改。但要注意:切到人工审核会停掉循环,切回全自动 / 半自动后还需要重新点「启动」。改之前想清楚,别在任务跑到一半时来回切。

十一、本章小结与下一步

最重要的一句话

「什么算做完」必须写进任务描述。界面没有单独的验收标准输入框,验收 Agent 就靠你这段描述判分。

三个最常见的误解,趁热澄清

到这里,你已经知道「发起任务之后系统做了什么」。下一章我们把镜头转向你自己:怎么把话说对——同样一件事,说法不同,AI 的产出质量天差地别。第 12 章会给你 100 多个可直接复制的提问模板。

下一章:提问的艺术(100+ 模板) 回看:自动运营:任务、轮次与验收 回看:软件功能的开发与修改

附录 A · 端到端时序全表

把「从点击到收到成品」的每一步摊开。失败会怎样一列,是这一表最值钱的部分。

#步骤触发者系统做什么你在界面看到什么大概耗时失败会怎样
1配置就绪你定运行模式、确认策略、配预算、建 Agent、开功能开关自动运营控制台、引导建项、功能管理一次性缺配置 → 启动被拦或任务不动
2新建任务你表单校验 → 写库 → 状态 pending任务管理列表多一行「待执行」秒级校验不过 → 弹错误提示,不入库
3等调度循环按排班表,下一轮选中该任务轮次页出现新轮次一个轮间间隔内循环未跑 → 一直 pending
4轮前预算检查循环查 AI 运行预算;≥80% 预警,超限熔断计费明细「预警 / 已熔断」-熔断 → 暂停循环 + 通知
5组装提示词系统拼任务描述 + 接力摘要 + 角色设定 + RAG + 优秀案例日志里可间接看到知识库引用秒级角色/RAG 缺失 → 用默认值兜底
6选择引擎系统任务级 > 角色级 > 项目默认 → loop/agent轮次页「引擎」列即时引擎未就绪 → 跳过该轮并记录
7执行一轮引擎loop 起子进程 / agent 进程内 LLM+ToolCall状态「运行中」,日志实时滚动分钟级(视任务)超时 → 强杀,进入下一轮(不算失败)
8计费入账系统按 token 单价折算,写计费明细 + 项目账本计费明细累计花费、输入/输出 Token轮末上游无 usage → 按长度估算(标注「估算」)
9生成交接班记录系统提取「目标/动作/未完成/下一步」存档日志「summary」标签轮末超长截断,不影响流程
10完成判定系统看输出末尾有无完成标记无直接入口,但从轮次状态推断即时无标记 → 下一轮继续(不是失败)
11人工/敏感拦截系统红/黄通道 → 建人工节点,任务暂停等待通知中心「审批请求」;人工处理节点「待处理」等你超 SLA → 升级或降级(见附录 B)
12独立验收验收 Agent对照任务描述判定 pass / redo / reject验收记录页新增记录分钟级解析失败 → 降级 redo + 转人工复核
13结论流转系统pass→完成;redo→回队列;reject→升级人工任务状态与验收结论变化即时redo 超上限 → 转人工复核
14通知你系统按类型与优先级走站内/飞书/Telegram/移动审批通知中心 / 手机秒级渠道异常 → 降级为站内提示
15轮次推进循环sleep 间隔后进入下一轮;达 20 轮或全完成转 review轮次页轮次号递增间隔默认 60 秒调度损坏 → 从备份回退
16失败兜底系统1–2 次降级重试 → 第 3 次升级人工 → 超限告警退出兜底保护暂停横幅(控制台「项目已因兜底保护暂停」/详情页「自动运营已因兜底保护暂停」)-退出后需人工处理再「恢复」
17全完成空闲循环进入 free 等待,不消耗 LLM,按间隔再 review通知「项目已完成全部任务并空闲等待 N 轮」持续注入新信息 / 触发 review 可继续

附录 B · 「我的任务为什么没动」排查树

从上往下,一层层问自己。每一支都给了「怎么确认」和「怎么办」。

症状怎么确认怎么办
项目没启动 项目详情页头部状态不是「运行中」;项目状态可能是 paused / stopped 点「启动」或「恢复」
自动运营没开 自动运营控制台状态不是「运行中」,或卡片显示未启用 点「启动」;若被策略门槛拦住,先去确认执行策略
策略未确认 引导建项页「策略确认」显示「策略未确认」 去项目执行策略卡点「确认策略」「完成建项」,再启动
人工审核模式 运行模式显示「人工审核」 这是设计行为——循环不跑。要么手动触发任务,要么切回全自动/半自动再启动
任务在排队 运行轮次页有轮次在跑,但选中的是别的任务 正常。想更快:提时间片权重、提优先级、减任务数
任务自身被暂停 任务列表该行状态是「已暂停」 点该行的「恢复」
任务在「规划中」 任务是 eng / mod 类型,状态是「规划中 planning」 规划中的任务不参与调度。点「继续规划」或「继续修改」把向导走完
等待人工节点 人工处理节点页有「待处理」,且关联到该任务 去审批(确认完成 / 批准 / 移动审批)
预算熔断 计费明细显示「已熔断」;自动运营控制台「熔断:是」 补足预算 → 点「恢复」继续(页面引导指向「恢复」)
兜底暂停 控制台显示「项目已因兜底保护暂停」(项目详情页措辞为「自动运营已因兜底保护暂停」) 兜底是持久状态。查日志找连续失败原因,处理后在控制台点「恢复」继续(兜底暂停时不再引导去点已禁用的「启动」)
空闲等待 free 收到「已完成全部任务并空闲等待 N 轮」通知 不是故障。注入新信息或触发 review 重排任务即可继续
验收返工中 验收记录里该任务最近一条结论是「返工」 正常质量把关。看验收报告,必要时修改任务描述让标准更明确
引擎执行超时 轮次耗时接近「时限(秒)」,状态可能为超时 超时后自动进入下一轮(不算失败)。任务太大就拆分,或调大「时限(秒)」
连续失败退出 任务 fail_count 高,系统通知里有告警 降级重试→升级人工→告警退出。查日志定位根因(依赖缺失、权限不足等),处理后恢复
排查口诀

先看模式(人工审核?),再看开关(循环启动了吗?),再看钱(熔断了吗?),再看轮次(排到了吗?),最后看节点(在等你吗?)。九成的「任务不动」逃不出这五问。

附录 C · 引擎选择决策表

拿不准用哪个引擎时查这里。默认建议:不确定就用 loop。

任务特征推荐引擎原因风险
写代码、改代码、修 Bugloop需要真正读写文件、跑命令agent 做会只出「伪代码/片段」
构建、部署上线loop长时、多步骤、涉及环境agent 无法执行构建
跑测试并修复loop需要反复执行与验证agent 无法实跑
复杂多步骤工程任务loop长上下文、可迭代轮次多、花费高
查询一条信息agent快、便宜复杂任务会不堪重负
汇总 / 翻译 / 分类agent信息整合,无外部副作用需注意输出准确度
生成文案、邮件草稿agent内容生成为主对外发送仍需人工审核
基于知识库问答agent检索 + 生成,轻量知识库没料会答得空
调用外部接口 / 发通知 / 发邮件agent以工具调用为主写操作要人工审核
数据分析出报表agent整合 + 计算数据源未接则无数据
描述含糊、不确定loop(兜底)安全默认值,能力更强费用相对高
要交付一个能跑的东西loop软件交付必须 loop用 agent 会拿不到可用交付物
想先低成本探路agent 试跑,再切 loop先小成本验证方向要记得在正式交付前切回 loop
界面原文再强调一次

软件工程 / 软件修改类任务选中 Agent 智能体时弹的警告是:「Agent 引擎可能无法完成软件交付,仅适合简单项目,建议使用循环执行」。这不是客套话,是实打实的交付边界。

附录 D · 设计依据摘录(为什么这么设计)

下面每条都是从设计文档里摘的「意图」,配上人话解释。想深入了解的读者,出处文件在本节末尾。

设计点设计文档的意图人话解释
时间片 + 轮次制 「按『时间片 + 轮次制』将多任务轮流推进,保证每个任务周期性获得处理时间」 不让一个卡住的长任务拖垮全局;急的任务给更多片,大家轮流获得关注。
接力摘要(task_summary) 「每轮结束保存 task_summary(本轮目标/动作/未完成点/下一步),下一轮注入继续」 让 AI「睡一觉回来还记得干到哪」,支撑跨小时、跨天的长期运行。
完成标记驱动 「输出末尾出现 [Task finished] 标记 → 触发独立验收」 用一条明确信号决定「这一轮算不算干完」,避免「差不多」的模糊判定。
三权分立验收 「执行(员工 Agent)/ 验收(独立验收 Agent)/ 批准(负责人)三方分离,防止自审自批」 干活的和判分的不能是同一个 AI,否则质量没人把关。
review 轮 「定期让 AI 审视全局(git log、进度、预算、收益),重排任务集与时间片」 项目跑久了方向会偏,需要定期停下来重新看全局、重新排活。
free 空闲等待 「任务集为空或全完成时进入,只做常规检查、按间隔再 review,避免空转烧钱」 活儿干完了就歇着,别让 AI 为了「有事做」而空烧 token。
失败兜底三级 「第 1–2 次降级重试 → 第 3 次升级 → 超上限告警退出(通知 + 暂停循环,防烧钱)」 出问题先自救、再找人、最后停下来;绝不无限重试烧钱。
暂停不杀子进程 「pause 是当前轮执行完成后进入等待,不杀正在执行的子进程,避免丢上下文」 半路掐断会让 AI 忘记进度,所以停要停得「文明」。
只有全自动/半自动跑循环 「run_mode=full_auto/semi_auto 才启用 auto-ops;manual_review 不启用」 人工审核模式就是要人盯,不能背着人自动跑。

出处:以上分别摘自 wiki/TAD-v2/04-autoops-调度与轮次.md(模块一 1.1、模块四 4.4.3/4.4.4/4.4.6、模块五 5.4)与 wiki/TAD-v2/02-项目服务器执行引擎.md(模块二 2.1/2.4.3/2.4.7)。空转与兜底的原文另见 wiki/manuals/zy-engine/release/04-autoops调度与轮次/使用手册.md 第一节与第六节。